Nano Banana是一款领先的AI图像编辑器,通过简单的文本提示转换任何图像。
Nano Banana是由Google的Gemini Flash Image技术提供支持的先进AI图像编辑工具,通过智能多模态图像转换重新定义创意可能性,快速、高质量地实现图像编辑。
体验革命性的AI图像处理,快速生成专业内容。
nano banana google利用Gemini闪光图像和nana banana ai技术,提供革命性的AI图像处理服务。核心优势包括智能图像生成、一键风格转换、智能图像优化等。
使用Grok Video将想象转化为视频
Grok Video是一款AI视频生成工具,能够将任何图像转化为专业视频,无需编辑技能。其主要优点在于快速生成高质量视频,提供多种格式输出,支持自然语言控制,以及无创意限制。
自动提取和总结 arXiv 研究论文的 Python 工具。
该产品是一个 Python 脚本,利用 Gemini API 从 arXiv 获取和总结研究论文。它帮助研究人员、学生和爱好者快速提取关键信息,从而节省阅读冗长文献的时间。该工具不仅适合个体用户,还可以自动化日常的文献检索,提升研究效率。产品免费提供,易于安装和配置。
基于 Gemini 的 Colab 数据科学助手,可自动生成完整的 Colab 笔记本代码。
Data Science Agent in Colab 是 Google 推出的一款基于 Gemini 的智能工具,旨在简化数据科学工作流程。它通过自然语言描述自动生成完整的 Colab 笔记本代码,涵盖数据导入、分析和可视化等任务。该工具的主要优点是节省时间、提高效率,并且生成的代码可修改和共享。它面向数据科学家、研究人员和开发者,尤其是那些希望快速从数据中获取洞察的用户。目前该工具免费提供给符合条件的用户。
一个基于Gemini 2.0 Flash模型的Perplexity风格AI搜索引擎。
Gemini-Search是一个模仿Perplexity的AI搜索引擎,它利用了Google的Gemini 2.0 Flash模型和Google搜索API,能够提供实时的网络搜索结果和引用,帮助用户快速获取准确的信息。该产品的主要优点在于其快速的响应时间和清晰的用户界面,使其在信息检索方面具有很高的效率。该产品适用于需要快速获取信息的用户,如研究人员、学生和专业人士。产品目前是免费的,适合各种规模的用户使用。
利用Gemini API生成小型应用
Gemini Coder是一个基于Gemini API的项目,旨在通过一个简单的提示生成小型应用。该项目完全基于llamacoder,并使用了Next.js、Tailwind等技术栈。它允许用户快速创建应用,并且可以本地运行和测试。作为一个个人项目,它并非Google官方项目,但展示了利用先进API进行应用开发的潜力。
一个集成了Gemini多模态直播和WebRTC技术的单文件应用
Gemini Multimodal Live + WebRTC是一个展示如何构建简单语音AI应用的示例项目,使用Gemini多模态直播API和WebRTC技术。该产品的主要优点包括低延迟、更好的鲁棒性、易于实现核心功能,并且兼容多种平台和语言的SDK。产品背景信息显示,这是一个开源项目,旨在通过WebRTC技术提升实时媒体连接的性能,并简化开发流程。
一个展示Gemini 2.0原生音频能力的实验性文本编辑器
Voice Cursor是一个基于Gemini 2.0原生音频能力的实验性文本编辑器,它展示了如何将Gemini的新文本到语音API集成到文本编辑器中,以实现流畅、上下文的声音生成。这个项目不仅展示了Gemini 2.0的强大新功能,还提供了一个实际应用的示例,允许开发者和用户探索和利用这一新技术。产品背景信息包括Google Creative Lab的创新项目,旨在推动技术边界并提供新的交互方式。产品目前是免费的,主要面向开发者和技术爱好者,适合那些寻求创新解决方案以提高生产力和无障碍访问的个人或团队。
谷歌开发的AI模型,提供推理能力更强的响应。
Gemini 2.0 Flash Thinking Mode是谷歌推出的一个实验性AI模型,旨在生成模型在响应过程中的“思考过程”。相较于基础的Gemini 2.0 Flash模型,Thinking Mode在响应中展现出更强的推理能力。该模型在Google AI Studio和Gemini API中均可使用,是谷歌在人工智能领域的重要技术成果,对于开发者和研究人员来说,提供了一个强大的工具来探索和实现复杂的AI应用。
利用LLM读取源代码并提供问题解答
askrepo是一个基于LLM(大型语言模型)的源代码阅读工具,它能够读取Git管理的文本文件内容,发送至Google Gemini API,并根据指定的提示提供问题的答案。该产品代表了自然语言处理和机器学习技术在代码分析领域的应用,其主要优点包括能够理解和解释代码的功能,帮助开发者快速理解新项目或复杂代码库。产品背景信息显示,askrepo适用于需要深入理解代码的场景,尤其是在代码审查和维护阶段。该产品是开源的,可以免费使用。
自动化创建WordPress标准文章的插件
AIEntries是一个WordPress插件,利用Google的GEMINI人工智能和stability.AI,根据WordPress管理视图中的可配置参数自动化创建标准文章。它结合了多个免费API来确保内容质量,包括获取真实文章的News API、基于真实文章生成原创内容的Google Gemini API,以及根据AI生成文章标题生成文章特色图片的Stability AI。
与Chrome和Gemini Nano无缝协作的AI助手。
LocalhostAI是一款旨在提高用户生产力的AI助手应用。它与Chrome浏览器和Gemini Nano设备紧密集成,使用户能够利用先进的AI模型来提升工作效率。该产品的主要优势在于其内置的Chrome AI模型、支持离线使用、注重隐私保护、运行速度快且完全免费。
一键部署您的私人Gemini应用
TalkWithGemini 是一款支持一键免费部署的跨平台应用,用户可以通过这个应用与 Gemini 模型进行交互,支持图片识别、语音对话等多模态交互方式,提高工作效率。
将 Google Gemini 引入到 ComfyUI 中,用于生成提示词和对话
ComfyUI-Gemini 是一款将 Google Gemini 模型集成到 ComfyUI 中的插件。用户可以利用 Gemini 模型生成提示词、与之对话聊天,并且支持多模态输入如图像。该插件免费使用,提供隐式和显式两种 API Key 使用方式,适合个人和团队使用。
在Google搜索中集成Gemini和GPT-4的侧边栏
SidePanel for Gemini and GPT-4 Google Search是一个Chrome插件,它将Gemini和GPT-4与Google搜索无缝集成,使您能够在一个地方获得答案、见解和信息。它还通过使用GPT-4添加相关的网页结果,确保您获得最准确、最全面的信息。
Gemini API的指南和示例集合
Gemini API Cookbook是一个包含Gemini API使用指南和示例的集合,旨在帮助开发者快速上手并使用Gemini API。这些示例大多数是用Python编写的Colab Notebooks,可以直接在Google Colab中打开或下载到本地环境中运行。
Text to 3D的巨大飞跃,优化的Web应用,欢迎共享和学习。
Meshy-2是我们3D生成AI产品系列的最新成员,距离Meshy-1发布已经过去三个月。这个版本在Text to 3D领域有着巨大的飞跃,为3D对象提供更好结构的网格和丰富的几何细节。在Meshy-2中,Text to 3D提供了四种风格选择:真实、卡通、低多边形和Voxel,以满足各种艺术偏好并激发新的创意方向。我们提高了生成速度,不影响质量,预览时间约为25秒,精细结果在5分钟内完成。此外,Meshy-2引入了用户友好的网格编辑器,具有多边形数量控制和四边形网格转换系统,以提供更多3D项目中的控制和灵活性。Text to Texture功能经过优化,以更清晰的效果呈现纹理,速度提高一倍。Image to 3D的增强功能在2分钟内生成更高质量的结果。我们正在将重心从Discord转移到Web应用,鼓励用户在Web应用社区中分享AI生成的3D艺术。
© 2025 AIbase 备案号:闽ICP备08105208号-14